刚刚!Claude Fable 5,又拿第一了
刚刚!Claude Fable 5,又拿第一了Claude这次,真把AI编程榜单打出断层了!就在刚刚刷新的MirrorCode排行榜上,Claude Fable 5以64%的绝对成功率再次登顶。 排在第四的GPT-5.5更惨。不仅成绩只有10%,甚至还被自家前辈GPT-5.4按在地上摩擦。
搜索
Claude这次,真把AI编程榜单打出断层了!就在刚刚刷新的MirrorCode排行榜上,Claude Fable 5以64%的绝对成功率再次登顶。 排在第四的GPT-5.5更惨。不仅成绩只有10%,甚至还被自家前辈GPT-5.4按在地上摩擦。
其实 Codex 和 Claude Code 都支持切换模型,咱们直接用 DeepSeek-V4-Flash 来驱动它们就行,量大管饱、不用魔法、也不怕封号。而且现在 DeepSeek 官方已经做了原生适配,接入流程比以前简单多了。
8 月 3 日,阿里巴巴正式发布新一代基座大模型 Qwen3.8,总参数量 2.4 万亿,在编程(Coding)和专业办公(Cowork)方面能力大幅提升。今日放榜的权威三方榜单 Arena 中,阿里 Qwen 模型仅次于 Anthropic 的 Claude 系列,整体性能处于全球大模型第一梯队。。
「我明天要见心理咨询师,」一位居住在波士顿的年轻妈妈,正在规划第二天的行程,不过,这话她既不是说给丈夫听的,也不是说给孩子听的,而是说给 Claude 听的。「帮我捋一捋上次咨询之后我们聊过什么,有什么该拿出来说的。」
整个AI圈,都在为Opus 5沸腾!
最近有个挺有意思的对比实验,来自 Composio 团队。他们用同一个模型 Kimi K3,分别放进三个不同的 agent 框架(harness)里跑 ——Claude Code、Hermes 和 Kimi Code—— 一共测了 28 个完全相同的任务。
我们整理了最近半年来 OpenCode CEO Jay V 以及联合创始人 Dax Raad 近期在多档播客和访谈中的核心观点,试图还原一个完整的图景,一家开源公司究竟如何在巨头夹缝中找到自己的位置,以及他们怎么看待商业化和模型编排。
旧金山市中心有一条很窄的小巷,名字叫 Claude Lane,巷子里开着一家全年无休的咖啡馆。凌晨两点,顾客仍然可以进来买咖啡、连无线网络、打开电脑工作。到了工作日下午,店里的桌子经常全部坐满,有人只能把电脑放在膝盖上。
近日,一家公司员工爆料,其所在公司已与其他企业一道收到了美国政府指令,要求停止使用 Anthropic 旗下的产品、服务和模型。按照通知要求,公司将在 2026 年 8 月 31 日前完成全面清退,适用范围覆盖所有员工、承包商、应用程序、开发环境、云服务,以及代表公司开展工作的第三方。
Claude,开始对密码算法下手了。